原帖 | Jason | 2026-05-04 17:01 | 👍0 | 阅读约1
Gemma 4 开源了,这次是真能塞进手机
4 月初 Google 开源 Gemma 4,4 个尺寸一次放出来:
- E2B / E4B(有效 2B / 4B 参数):手机、树莓派、Jetson 都能跑,完全离线,自带视觉和音频输入
- 26B MoE(实际激活 3.8B):消费级显卡能跑,速度快
- 31B Dense:单张 H100,目前开源模型综合排名第 3(26B 排第 6,比体量大它 20 倍的开源对手都强)
我想重点说说"能塞进手机"这件事为什么重要。过去做手机端 AI App 是个很憋屈的活——要么塞个 1B 的小模型进去,能力差得离谱;要么只能调云 API,离线场景全废、隐私问题让客户反感。
Gemma 4 的 E2B/E4B 是我看到第一个真的在手机上能跑得动、能力又过得去的开源多模态模型,原生支持 140 多种语言、上下文 128K、function calling 直接训练在里面。
什么意思?意味着接下来一年你会看到一波
"完全离线的 AI 翻译 App"
"完全离线的扫描总结 App"
"完全离线的语音助手 App"
这些以前都是大厂闭源 SDK 才能做的事,现在 Apache 2.0 许可,谁都能拿去商用。
最简单的尝鲜路径是装 Ollama,一行 ollama run gemma4,本地跑起来。
或者直接去 Google AI Studio选 gemma-4-31b-it 在线对话,免费。
相关笔记